V5.0

[随波逐流]OCR识别工具 使用说明书

截图即识 · 本地离线 OCR · 表格 / 条码 / 翻译 / 水印 / 双层 PDF / 批量转换 一体化的桌面效率工具

一、软件简介

随波逐流 OCR 识别工具是一款免费、免安装的 Windows 桌面效率工具,常驻系统托盘、随叫随到。屏幕上看到的文字,框一下就能变成可编辑文本——无论是网页文章、PDF 报告、表格单据,还是二维码、代码截图,统统一键识别。

  • 离线引擎,数据不出电脑:内置 本地识别核心,不联网也能识别,中文与中英混排效果好,敏感内容更放心。
  • 一站集成,不再东拼西凑:识别之外,翻译、整理、缩进、替换、水印、压缩、取色、图床全在这一个窗口里,装一个顶一堆小工具。
  • 识别只是开始:结果集中在主文本框中,直接编辑、翻译、排版、导出 txt,识别到的内容马上就能用。

默认使用本地离线引擎;也可在「配置」中填入百度 API Key,一键切换在线识别(适配离线效果不佳的特殊场景)。

 

和主流OCR工具做个对比

功能 本程序 V5 Umi‑OCR PandaOCR TextIn Text‑Grab NormCap ShareX 天若OCR
截图与标注
截图热键 / 全局截图 ✓ ✓ ✓ — ✓ ✓ ✓ ✓
截图标注 (形状/文字/马赛克) ✓ — — — — — ✓ ✓
序号标注 (圆底数字递增) ✓ — — — — — ✓ —
截图贴图 (钉屏) ✓ ✓ ◐ — ✓ — ✓ —
忽略区域 (免误识别) ✓ ✓ — — — — ◐ —
滚动截图拼长图 ✓ ◐ — — — — — —
识别核心
离线 OCR 引擎 ✓ ✓ ◐ —(云端) ✓ ✓ — ◐
多语言识别 ✓ ✓ ◐ ✓ — ◐ — ◐
超长/超宽图分块识别 ✓ ◐ — ✓ — — — —
竖排/多栏版式还原 ✓ — — ✓ — — — —
GPU 免配置加速 ✓ ◐ — — ✓ — — —
表格识别 → Excel ✓ ✓ — ✓ — — — ◐
二维码 / 条码识别 ✓ ✓ ✓ ◐ — ◐ ✓ ✓
二维码 / 条码生成 ✓ — — — — — ✓ —
文档与效率工具链
双层可搜索 PDF ✓ ✓ — ◐(云端收费) — — — —
PDF 批量转 TXT/DOCX+自动整理 ✓ — — ◐(云端) — — — —
PDF 压缩 / 加水印 / 转 Word ✓ — — ✓ — — ◐ —
批量图片识别导出 ✓ ✓ ◐ ✓ — — ✓ ◐
翻译 ✓ ✓ ✓ ◐ — — — ✓
✓支持   ◐部分支持/需联网或插件   —不支持 

 

三步上手

  1. 启动程序(默认最小化到托盘或直接显示主窗口)。
  2. 按 F8(默认文字识别快捷键),屏幕变暗后按住鼠标左键框选要识别的区域,松开即自动识别。
  3. 识别结果出现在主文本框中,可直接编辑、复制、导出;按 F7 仅截图不识别。
识别过程中按 Esc 可随时取消框选。
启动程序 按 F8 框选屏幕区域 自动识别 编辑 / 翻译 / 导出 识别过程中随时按 Esc 取消框选
图 1 · 三步完成一次识别

二、软件特色

① 本地离线识别
内置 识别离线引擎,断网照样识别,中文 / 中英混排效果好,完全免费不限量。
② 超长截图
滚动截图自动拼接;数千像素高的超长图自动分块识别、去重合并,一次出完整文本。
③ 表格识别
框选表格直接还原为Excel 表格,保留行列结构。
④ 多条码识别
一次框选可同时识别画面中的多个二维码 / 条形码,支持 QR、Data Matrix、PDF 417、EAN、Code 系列等 21 种码制(详见下表)。
⑤ PDF / 图片压缩转换
PDF 转 DOCX、PDF 四档质量压缩;图片批量压缩(保持原格式 / JPEG / PNG、可限宽)。
⑥ 屏幕取色
吸取屏幕任意位置颜色,返回颜色值,设计 / 前端取色利器。
⑦ 在线翻译
中英互译一键完成:长文自动分段、多引擎自动兜底,译文单独成框不混排。
⑧ 文本整理
一键排版:合并 OCR 断行、去字间空格、列表项独立成段、去除重复行,还支持多步撤销。
⑨ 图片水印
文字水印 7 项参数全可调(颜色 / 透明度 / 角度 / 间距 / 字号 / 平铺或单个 / 玻璃样式)。
⑩ 上传图床
图片一键上传免费图床并返回外链,发帖、分享、写文档直接引用。
⑪ 双层可搜索 PDF
扫描版 PDF 外观不变,叠加一层可搜索、可复制的文字——转出来的文件在 Word、浏览器里都能直接选中文字。
⑫ PDF / 图片批量转换
整个文件夹的 PDF 一起转 DOCX(默认、宋体 12 磅)或 TXT,电子版直取文字层秒出、扫描件自动 OCR 兜底;几十张图片批量识别导出 TXT / MD / CSV。
⑬ 截图标注全套
矩形 / 椭圆 / 箭头 / 画笔 / 荧光笔 / 文字 / 马赛克,工具选中后粘滞可连续绘制;序号徽章点击自动递增;Ctrl+拖拽框忽略区域防误识;截图可贴图钉屏对照。
⑭ 多语种识别
简体中文、繁体中文、英文、日文内置同一离线模型免下载;韩语等更多语种在配置中按需下载(约 10MB,一次下载永久离线可用)。

特色功能详解

  1. 文字识别——50+ 语言、横竖排自动识别。支持 50 余种语种文本解析,覆盖中英日韩、多语种欧洲语言、小语种及部分少数民族文字;自动判断文本排版方向,横向、竖排文字无需手动切换模式、无需提前矫正图片,轻微模糊、反光、倾斜的素材也能精准识别。追求更高精度可取消勾选「本地识别」切换百度在线接口(Key 自备);
    竖排繁体书法识别
    竖排繁体书法识别
    竖排日文识别
    竖排日文识别
    多语种识别
    多语种识别
    手写便签识别
    手写便签识别
    多语言按需下载(配置-OCR 引擎)
    多语言按需下载(配置-OCR 引擎)
    有独显的机器自动走 GPU 加速,没有也流畅。
  2. 全能截图——长图拼接 + 标注贴图一站式。勾上「滚动截图」后页面滚到哪拼到哪,长图自动接起来,配合超长图自动分块识别,多长的图都能吃下;拼接处有重复,「段落去重」顺手清掉。矩形、椭圆、箭头、画笔、荧光笔、文字、马赛克一应俱全;「序号标注」点击即放圆底数字徽章、自动递增、可拖动缩放,写步骤图省事;「忽略区域」框住水印头像防误识;「贴图」
    截图标注工具(矩形/椭圆/箭头/序号…)
    截图标注工具(矩形/椭圆/箭头/序号…)
    滚动截图进行中
    滚动截图进行中
    滚动截图自动拼接结果
    滚动截图自动拼接结果
    把截图钉在屏幕上对照抄参数。
  3. 条码识别与生成——全码制覆盖、批量解析。覆盖 Code 128、Code 39、EAN-13、EAN-8、UPC-A、UPC-E、ITF、Codabar 及 QR Code、PDF 417、Data Matrix、Aztec 等;支持一图多码一次识别全部输出;对拍照畸变、轻微倾斜、反光、噪点、局部遮挡自动做图像预处理增强;识别结果输出原始码数据,方便对接业务校验、数据录入与批量解析;
    拍照反光条码识别
    拍照反光条码识别
    Data Matrix 识别
    Data Matrix 识别
    MaxiCode 识别
    MaxiCode 识别
    多码混合一次识别
    多码混合一次识别
    右键菜单生成条码
    右键菜单生成条码
    支持的条码类型
    支持的条码类型
    支持批量图片解码并导出结果。
  4. 表格识别——图片一秒生成可编辑 Excel。自动定位图片内表格,还原行列、合并单元格结构,拍照、扫描件、截图均可识别,
    表格识别——图片一秒变可编辑 Excel
    表格识别——图片一秒变可编辑 Excel
    日文竖排翻译
    日文竖排翻译
    韩文翻译
    韩文翻译
    导出后无需手动录入排版。
  5. 在线翻译——识别即翻译。可对接识别后的文字直接翻译,省去复制粘贴;支持批量文本翻译,
    在线翻译
    在线翻译
    快速完成资料、文档语种转换。
  6. 文本整理——识别即成稿。「自动整理」把一行一断的原始结果合并成完整段落;「段落去重」专治滚动长图衔接处的重复内容;「自动缩进」管首行格式。三个勾全开,
    文本整理——断行合并成段落
    文本整理——断行合并成段落
    多语种长文翻译
    多语种长文翻译
    右键文本整理
    右键文本整理
    识别结果基本不用再动手改。
  7. 图片水印——文字水印防盗用。水印内容、透明度、大小与排布方式均可自定义,支持全屏平铺与角落单水印,
    水印配置(文字/透明度/角度/平铺)
    水印配置(文字/透明度/角度/平铺)
    桌面贴图(钉屏对照)
    桌面贴图(钉屏对照)
    保护图片版权。
  8. PDF 工具——常用处理一站集成。批量转换:整个文件夹的 PDF 一起转 DOCX 或 TXT(默认 DOCX、宋体 12 磅),自带文字层的电子版直接秒出,扫描件自动逐页 OCR 兜底;同一页签还有双层可搜索 PDF(外观不变、全文可搜可复制)与一键压缩,
    PDF 批量转换(DOCX/TXT/双层/压缩)
    PDF 批量转换(DOCX/TXT/双层/压缩)
    转换选项(自动整理/段落去重/缩进)
    转换选项(自动整理/段落去重/缩进)
    批量转换进行中
    批量转换进行中
    双层可搜索 PDF 页签
    双层可搜索 PDF 页签
    适配存档、上传、发布、打印场景。
  9. 图片处理——批量识别 + 批量压缩。批量图片识别:整个文件夹的图一次跑完,进度实时可见、中途能停,跑完按单文件导出 TXT / MD / CSV / DOCX,离线引擎本地跑、敏感单据不出电脑;批量图片压缩:自定义压缩质量,肉眼画质损失很小前提下大幅减小体积,
    批量图片识别——一文件夹的图一次跑完
    批量图片识别——一文件夹的图一次跑完
    批量图片压缩
    批量图片压缩
    压缩后可打包下载。
  10. 屏幕取色——一键取色。拾取屏幕任意位置颜色,获取十六进制、RGB 色值并支持复制色号,UI 设计、调色、
    屏幕取色
    屏幕取色
    取色结果(HEX/RGB 色值)
    取色结果(HEX/RGB 色值)
    网页开发快速取用。
  11. 智能版面整理——文档级还原,不止于文字。识别结果自动还原文档版面:两栏 / 多栏按正确阅读顺序输出,跨栏大标题不拆碎;竖排文字(古籍、题字、对联)从右到左逐列还原,竖排标点多配置精读自动挽回;勾选「剔除页眉页脚」自动剔除书页顶 / 底部的页眉页码;勾选「标题层级」(配置 → 整理设置)自动加 Markdown 标题前缀,一键导出结构化 .md 文档;表格识别结果以 Markdown 表格并入文本框、另存 Excel 双格式输出。
还有更多功能等待您的发现。

支持的条码类型(共 21 种)

1D 商品码1D 工业码2D 码
UPC-ACode 39QR Code
UPC-ECode 93Data Matrix
EAN-8Code 128Aztec
EAN-13CodabarPDF 417
UPC/EAN Extension 2/5ITFMaxiCode
BarcodeRSS-14
RSS-Expanded
超市商品条码(EAN-13 / UPC-A)、快递单(Code 128)、名片二维码(QR Code)、火车票 / 单据上的 PDF 417 等日常条码全覆盖。
详见下文按钮逐个介绍。

三、软件界面

区域说明
顶部按钮栏25 个功能按钮(鼠标悬停有浮框提示、高亮反馈):识别类 → 文本处理 → 文件 → 工具 → 系统。最左侧是软件图标,按住可拖动窗口。
主文本框识别结果与编辑区,支持多步撤销(最多 20 步)。点击「显示/隐藏文本框」可收起整窗。
译文框点击「在线翻译」后在右侧出现,含「复制 / 导出 / ✕ 关闭」。
底部勾选栏9 个功能开关(详见第八节),展开文本框时显示。
更新提示行有新版本时在文本框下方显示红色提示与「升级」按钮。
系统托盘点 ✕ 关闭仅隐藏到托盘,双击托盘图标或按 Ctrl+F1 恢复。
窗口无边框:除按钮外,顶部留白区域与软件图标都可按住拖动窗口。
收缩态工具栏——平时只是一条小工具栏
收缩态工具栏——平时只是一条小工具栏
展开态主窗口(识别结果、标注与勾选栏)
展开态主窗口(识别结果、标注与勾选栏)

四、按钮逐个介绍(从左到右)

按主界面上从左到右的实际排列顺序逐个介绍(序号即从左数第几个):

从左数按钮功能说明
第 1 个文字识别核心功能:框选屏幕区域识别为文字(快捷键 F8),默认本地离线引擎。
第 2 个屏幕截图仅截图不识别(快捷键 F7),截图进剪贴板。
第 3 个条码扫码框选二维码 / 条形码,解码结果直接写入文本框。
第 4 个表格识别框选表格区域输出 Excel 表格。
第 5 个在线翻译中英互译,译文显示在右侧译文框;长文自动分段、多引擎自动兜底(见第六节图 4)。
第 6 个首行缩进按「配置 → 缩进量」为段落首行加缩进(默认 2 全角空格)。
第 7 个文本整理一键排版:合并 OCR 断行、去字间空格、列表项独立成段、去除重复行。
第 8 个文本替换弹出查找 / 替换对话框,对文本框内容批量替换。
第 9 个撤销多步撤销(最多 20 步):替换、整理、清空、缩进等操作都能回退。
第 10 个清空清空文本框内容;误清可点「撤销」找回。
第 11 个复制一键复制文本框全部内容到剪贴板。
第 12 个粘贴先清空文本框,再贴入剪贴板内容——文字、截图均可(与右键粘贴的光标插入不同)。
第 13 个上传图床上传图片到免费图床并返回外链,方便发帖分享。
第 14 个导入把 .txt(自动识别编码)、.docx 或图片文件导入文本框;旧版 .doc 请先转存 .docx。
第 15 个导出 把文本框全部内容保存为 txt / Markdown(.md)文件,图片保存为图片文件。
第 16 个水印按「配置」中的参数给图片加水印(文字 / 颜色 / 透明度 / 角度 / 间距 / 字号 / 平铺或单个 / 玻璃样式)。
第 17 个PDF 工具四个页签:PDF 转 DOCX(转 Word 可编辑文档)、PDF 压缩(四档质量)、双层 PDF(外观不变叠加可搜索可复制文字层)、批量转换(整个文件夹转 DOCX / TXT / 双层 PDF,自动整理,扫描件自动 OCR 兜底)。基于内置 Ghostscript,无需另装组件。
第 18 个图片压缩批量压缩图片:保持原格式 / JPEG / PNG、压缩比滑块、可限定最大宽度。
第 19 个批量图片识别选一个文件夹,几十张图片一次跑完:进度实时可见、中途可停止;勾选「收缩时隐藏」后最小化不打扰工作。结果按单文件导出 TXT / Markdown / CSV(Excel 可开)。
第 20 个屏幕取色吸取屏幕任意位置颜色,返回颜色值,做设计 / 写网页常用。
第 21 个配置打开配置窗口:常规(启动最小化、快捷键、缩进量)、整理设置(段落去重、标题层级)、百度联网识别、水印全套参数、OCR 引擎(识别语言、GPU、阈值等),分五组排列。
第 22 个赞赏打开「赞赏作者」窗口,扫码支持作者。
第 23 个帮助打开在线帮助教程页(http://www.1o1o.xyz/bo_ocr.html)。
第 24 个更新手动检查新版本;发现新版本时文本框下方出现红色提示行与「升级」按钮。
第 25 个显示/隐藏文本框收起 / 展开文本区与底部勾选栏,让窗口缩成一行按钮,不遮挡工作区。
第 26 个✕ 关闭隐藏主窗口到系统托盘(并非退出),按 Ctrl+F1 或双击托盘图标恢复。
最右侧的 ✕ 之后没有其他按钮;最左端的软件图标(不是按钮)按住可拖动整个窗口。

五、识别功能

功能用法与说明
文字识别 F8框选区域 → 识别为文本。勾选「本地识别」走离线引擎;取消勾选则调用百度在线接口(需在配置中填 API Key)。含智能排版:自动合并断行、去重复行、按语种补空格,并自动过滤低置信度的碎字噪声(保留长文本,不误删正文)。
多栏 / 竖排还原两栏、多栏文档按「左栏读完读右栏」的正确阅读顺序还原,跨栏大标题自动先于正文输出;竖排文字(古籍、对联、题字)按从右到左逐列还原,竖排标点通过多配置精读自动挽回,不会整篇丢句读。
屏幕截图 F7仅截图不识别,图片保存到剪贴板。截图后可用工具栏「贴图钉屏」把选区钉在桌面上。
截图标注框选后可在选区内标注:矩形 / 椭圆 / 箭头 / 画笔 / 荧光笔 / 文字 / 马赛克。工具粘滞——选中后可连续绘制,直到切换工具或再次点击取消;序号标注点击放置圆形数字徽章、自动递增,可拖动移动、悬停滚轮缩放,撤销后序号自动回退。Ctrl+拖拽可框选忽略区域(红框标出,识别时剔除水印头像等)。标注会一并进入 OCR、保存与复制结果。
贴图钉屏截图工具栏「贴图」按钮:把选区钉成置顶无边框小窗——按住拖动移动、滚轮缩放(光标位置不动)、双击或右键关闭,可同时钉多张。照着参考图抄参数、对照录入时很好用。
多语言识别「配置 → OCR 引擎 → 识别语言」选择语种:简体中文+英文、繁体中文、日文内置同一离线模型免下载;韩语等更多语种首次选用需联网下载模型(约 10MB,一次下载永久离线可用)。
条码扫码框选二维码 / 条形码,识别结果直接写入文本框。
表格识别框选表格区域:结果以 Markdown 表格插入文本框(可直接复制进 Word / 笔记软件),同时弹出保存对话框另存 Excel(.xlsx)文件,双格式一次拿到。
滚动截图(勾选)开启后支持滚动拼接:多次截图自动上下拼接成超长图再识别。软件对超高长图(数千像素高)会自动分块识别并合并结果,无需手工切图。
超长截图 分块 1 ≤1500px 分块 2 与块 1 重叠 200px 分块 3 与块 2 重叠 200px 逐块本地 OCR 坐标还原对齐 重叠区去重 智能合并 完整文本 写入文本框 数千像素高的滚动拼接长图 → 自动切分 → 逐块识别 → 去重合并,全程无需手工处理
图 3 · 超高长图自动分块识别

六、文本处理

功能用法与说明
在线翻译 把文本框内容中英互译,译文显示在右侧译文框。内置多个翻译接口。
文本整理一键排版:合并 OCR 断行、清除 CJK 字间空格、列表项独立成段、去除重复行(数字归一化对比);保留段落间距(空行),一级 / 二级列表自动分级缩进。
标题层级(配置勾选)在「配置 → 整理设置」勾选「标题层级」后,识别时按行高聚类自动给标题行加 Markdown # / ## 前缀,配合「导出 → Markdown」可直接得到带层级的 .md 文档(导入 Typora、Obsidian 等笔记软件即为标准标题)。
首行缩进按「配置 → 缩进量」所选单位(默认 2 全角空格)为段落首行加缩进。
文本替换弹出「查找 / 替换」对话框,对文本框内容批量替换。
撤销多步撤销(上限 20 步):替换、整理、清空等操作均可回退。
复制 / 粘贴按钮「粘贴」= 先清空文本框再贴入剪贴板内容(文字或图片均可);右键「粘贴」= 在光标处插入,不动已有内容(详见第八节)。
清空清空文本框(可撤销)。

七、文件与图片工具

功能用法与说明
导入把 .txt(自动识别编码)、.docx、常见图片导入文本框;旧版 .doc 请先转存 .docx。
导出把文本框内容保存为 txt 或 Markdown(.md)文件——勾选「标题层级」后导出的 .md 自带 # 标题结构,可直接导入笔记软件。
上传图床把图片上传到免费图床并返回外链;右键菜单也可对选区图片使用。
水印对图片加水印:文字、颜色、透明度、角度、间距、字号、平铺 / 单个模式、玻璃磨砂样式均可在「配置」中调整(默认文字「随波逐流版权所有」、红色、50% 透明、-40°)。
图片压缩批量压缩:选输入路径与输出目录,支持保持原格式 / JPEG / PNG,压缩比滑块、限定最大宽度。
PDF 工具四个页签:PDF 转 DOCX;PDF 压缩(四档质量);双层 PDF——逐页识别并叠加不可见文字层,外观不变、可搜索可复制;批量转换——整个文件夹转 DOCX(默认、宋体 12 磅)/ TXT / 双层 PDF,勾选「自动整理」连段落都排好,自带文字层的电子版秒出、扫描件自动逐页 OCR 兜底。基于内置 Ghostscript,无需另装组件。
批量图片识别选文件夹批量识别:进度实时、中途可停、识别中可最小化;结果合并导出 TXT / Markdown / CSV(Excel 可开)。离线引擎本地运行,整批单据不出电脑。
屏幕取色框选或点击屏幕任意位置取色,返回颜色值。
配置 / 更新 / 帮助 / 赞赏配置见第九节;更新检查新版本;帮助打开在线教程页。

八、功能开关(底部勾选栏)

开关作用
窗口置顶主窗口始终保持在最前,不被其他窗口遮挡。
本地识别勾选 = 本地离线 OCR;取消 = 百度在线识别(需配置 Key)。
追加识别新识别内容追加到文本框末尾,不清空已有内容。
自动整理识别完成后自动执行「文本整理」。
自动缩进识别完成后自动执行「首行缩进」。
剔除页眉页脚识别书页 / 文档扫描件时,按版面位置自动剔除页顶 / 页底带内的页眉、页脚、页码(如「第 12 页」「- 3 -」),正文不受影响;滚动长图不适用。配合「自动整理」使用,转档文档更干净。
滚动截图启用滚动拼接长图模式。
自动水印识别完成后自动按配置给图片加水印。
开机自启通过启动项快捷方式实现开机自动运行;取消勾选即移除。
除「滚动截图」为当次会话有效(关闭或重启后自动复位)外,其余开关状态与配置项自动保存,下次启动保持不变。「段落去重」「标题层级」在「配置 → 整理设置」分组中勾选,勾选后识别 / 整理时自动生效。

九、右键菜单

在主文本框上点右键:

菜单项说明
复制 / 剪切 / 粘贴常规剪贴板操作。注意:右键「粘贴」是光标处插入,与顶部按钮「粘贴」(先清空再贴)不同。
导入文件到文本框 / 导出文本框内容同顶部「导入 / 导出」按钮。
截图文字识别 / 截图表格识别临时框选识别,不打断当前内容。
百度文字搜索 / 必应文字搜索把选中文本直接送去搜索引擎。
图片上传图床上传文本框中的图片并复制外链。
二维码 / 条码生成二级菜单选码制(QR Code、Data Matrix、Code 128、EAN-13 等),对选中文本(未选中则取全文)生成二维码 / 条码图片,可直接粘贴到聊天或文档。

十、配置窗口

配置窗口按功能分为五组:

1、常规(启动 / 快捷键 / 缩进)

配置项说明
启动时最小化勾选后启动驻留系统托盘、不弹主窗口,适合开机自启常驻场景。
OCR 快捷键 / 截图快捷键默认 F8 / F7,可改成 ctrl+f1、ctrl+alt+o 等组合。
缩进量首行缩进的单位(默认 2 空格全角)。

2、整理设置(段落去重 / 标题层级)

配置项说明
段落去重勾选后,识别完成与手动「文本整理」时自动执行整块重复段落去重——专治滚动长图衔接区重复内容。注意:歌词等合法重复也会被删,请酌情勾选。
标题层级勾选后,识别时按行高聚类给标题行自动加 Markdown # / ## 前缀,配合「导出 → Markdown」得到带层级的 .md 文档。

3、百度联网识别(仅未勾选「本地识别」时生效)

API Key / Secret Key使用百度在线识别时必填。

4、水印

配置项说明
水印文字 / 颜色 / 透明度 / 角度 / 间距 / 字号水印内容与样式,颜色点选色器选取(默认颜色为灰色 #808080)。
平铺模式tile = 平铺整图;single = 图片中央单个水印。
玻璃样式水印文字带磨砂半透明描边,更美观且不遮挡正文。

5、OCR 引擎(本地识别)

配置项说明
识别语言简体中文+英文、繁体中文、日文内置同一离线模型免下载;韩语等更多语种按需下载(约 10MB,一次下载永久离线可用)。
置信度阈值低于阈值的结果被丢弃。改小可多认出模糊文字但易出错(默认 0.5)。
方向纠正识别横排 / 180° 倒转文本(默认开)。
边长上限(px)送入识别引擎前图片最长边的缩放上限(默认 2000)。
计算模式自动探测(推荐,有独显自动走 GPU)/ 强制 CUDA / 强制 DirectML / 仅 CPU。
窗口底部有「默认设置」一键还原与「保存」按钮;所有配置自动保存,下次启动保持不变。

十一、快捷键一览

快捷键功能
F8文字识别(框选即识,可在配置中修改)
F7屏幕截图(仅截图,可在配置中修改)
Esc取消当前框选 / 截图
Ctrl+F1从托盘恢复主窗口
Ctrl+左键拖拽截图时框选忽略区域(识别时剔除),可添加多个
Ctrl+Z截图标注时撤销上一步标注 / 徽章

十二、常见问题

Q1:识别结果乱码 / 排版乱?

先点「文本整理」尝试自动修复;长图请确认已勾选「滚动截图」或使用滚动拼接,超高长图软件会自动分块处理。截取区域尽量贴合文字、避免过小的字号。

Q2:翻译失败或译文就是原文?

软件已内置多引擎级联与坏结果自动重试。若仍失败多为网络问题(部分引擎需要能访问外网),稍后重试即可;提示信息会写入日志。

Q3:程序关不掉了?

点 ✕ 是「隐藏到托盘」而非退出;双击托盘图标或按 Ctrl+F1 恢复后再从托盘图标右键退出。

Q4:出了问题怎么反馈?

程序目录下的 logging.log 记录了本次运行的全部信息(每次启动自动清空重建),反馈问题时请附上该文件。

Q5:在线识别报错?

检查配置中的百度 API Key / Secret Key 是否正确、账户是否有余额;不使用在线识别时保持「本地识别」勾选即可,完全免费离线。

Q6:日语 / 韩语识别不了?

到「配置 → OCR 引擎 → 识别语言」切换语种。简体中文、繁体中文、日文已内置同一离线模型,选中即用;韩语等更多语种首次选用会提示联网下载模型(约 10MB),下载一次永久离线可用。识别不出内容时会有空结果提示,请检查语言选择是否与图片一致。

Q7:扫描版 PDF 转出来能复制文字吗?

能。用「PDF 工具 → 双层 PDF」生成的文件外观不变,底层带可搜索、可复制的文字层;整个文件夹的 PDF 用「批量转换」页签一次转完(DOCX / TXT / 双层 PDF 可选,默认 DOCX)。

十三、关于本软件

  • 软件名称:[随波逐流]OCR识别工具
  • 在线帮助 / 最新版本:http://www.1o1o.xyz/bo_ocr.html
  • 本软件为免费软件,如果觉得好用,欢迎点「赞赏」支持作者。
  • 免费声明:本软件为永久免费软件,所有功能均可免费使用,不收取任何费用。如遇第三方以本软件名义进行收费售卖,均与本项目无关,请提高警惕、谨防受骗,下载请认准官方下载地址。
  • 官方唯一地址:随波逐流安全信息网 1o1o.xyz;下载地址:http://www.1o1o.xyz/bo_ocr.html
  • 持续更新:本工具依托 AI 辅助开发,大型项目持续迭代会产生较高 Token 开销,个人维护压力较大。若工具对您有所帮助,欢迎自愿赞助支持持续更新——赞助完全自愿,不付费不影响软件全部功能使用。
  • 这款工具从个人自用版本迭代至今,所有优化升级均来自真实用户反馈。始终坚持干净、免费、高效、无套路的初衷——不打扰、不收割、不泄露。